AI风向

【🔥突发】4TB语音数据泄露:4万AI工人的身份被打包出售,合成语音攻击正式爆发

4TB语音档案 + 政府证件 + 自拍照 = 完美语音克隆三角。攻击者要的不是一个密码,而是能随时冒用的"声音指纹"。Lapsus$这次泄露的数据,让任何人花15美元就能冒充他人——而这场灾难的受害者,恰恰是帮AI学会听说的那批人。

事件回顾

2026年4月4日,Lapsus$勒索组织在其泄密站点公布了Mercor公司的内部数据。泄露规模约4TB,涉及超过4万名AI训练承包商的敏感个人信息。

这批数据不是普通的简历或联系方式。Mercor的承包商入职流程要求三项核心材料:

  1. 政府签发的身份证件(护照或驾驶证扫描件)
  2. ** webcam自拍**(带时间戳的人脸照片)
  3. 坐姿语音录音(在安静房间内朗读指定内容,平均2-5分钟)

三项数据,同一个人,同一条数据库记录。这正是高保真语音克隆的标准输入。

《华尔街日报》2026年2月曾报道,市面上现成的语音克隆工具仅需约15秒干净语音即可生成高质量克隆。而Mercor的泄露录音平均时长2-5分钟,录音环境为录音棚级别静音——远超攻击阈值。

为什么这次泄露不同以往

过去十年,数据泄露属于两大类别之一:

  • A类:呼叫中心被攻击,录音泄露但无法关联到具体身份
  • B类:身份证件贩子泄露证件和自拍,但没有任何语音数据

Mercor打破了这一边界。语音生物特征 + 实名证件 + 人脸照片,三者首次在同一批次数据中同时出现。这意味着:

攻击者同时拥有克隆所需的声音模板证明"我是我"的凭证。以往需要社会工程学才能收集的信息,现在被一次性打包提供。

攻击者能用这些数据做什么

以下威胁模型均有先例可循,并非理论推演:

1. 银行声纹验证绕过

多家美国和英国银行仍以声纹作为双因素之一。攻击者用克隆声音朗读挑战语句即可通过音频验证,只剩密码问题——而密码信息往往同样来自泄露数据。2024年香港Arup公司员工在伪造多方视频会议中被诈骗约2500万美元,使用的正是公共影像素材构建的深度伪造。Mercor数据提供的是更高质量的"公共素材替代品"。

2. 冒充员工骗取雇主

致电受害者的HR或财务部门,以其声音要求转薪、汇款或解锁工作站。Krebs on Security档案记录了2023年以来超过24起已确认案件。

3. 保险理赔诈骗

Pindrop数据显示,2025年合成语音攻击同比增长475%,针对保险呼叫中心。汽车、寿险、伤残险是主要目标,因其主要通过电话受理。

4. 亲情诈骗

FBI互联网犯罪投诉中心(IC3)数据显示,2026年全年60岁以上受害者损失总额达23亿美元。增速最快的类别是紧急冒充电话——诈骗者以合成声音声称亲属处于困境需要紧急汇款。

我们能学到什么

1. 把语音样本当作不可更改的密码

语音生物特征无法像密码那样"更改"。一旦泄露,攻击者可无限使用。处理方式与对待泄露密码相同:假设它已被滥用,并主动限制其解锁能力。

2. 主动清除各平台的声纹注册

Google Voice Match、Amazon Alexa Voice ID、Apple Personal Voice、银行声纹登录——现在就去设置中删除并重新录制。新录音尽量选择与泄露样本不同的声学环境。

3. 向银行书面要求禁用声纹验证

以邮件形式要求银行将声纹从主要验证因素中移除,要求APP令牌或硬件密钥配合知识问题的多因素认证。大多数银行允许opt-out,但很少主动宣传。

4. 建立家庭暗语

与家人和财务处理人约定一个从未在录音或聊天中提及的短语。若来电要求转账,该暗语是必检项。这是成本最低、最有效的防御手段。

识别合成声音的取证清单

以下是声学取证专家拿到音频样本时的第一轮检查项——即便感知质量很高,合成语音也往往在这些维度露出破绽:

特征 真实语音 合成语音常见问题
呼吸模式 在可预测位置吸气 跳过或位置错误
微观抖动 声带振动有微小不规则 毫秒级过于干净
共振峰轨迹 口腔物理运动路径自然 跨越声道时出现不可能的捷径
房间混响 全程一致 干湿混音不一致
韵律变化 音高和能量方差自然 方差过窄,呈"平板"感
语速变化 内容驱动,有快有慢 长篇保持节拍器般稳定

行动建议

今天就能做的3件事:

  1. 检查自己是否曾是Mercor承包商 → 访问 haveibeenpwned.com 或类似平台核查
  2. 注销所有非必要的声纹注册 → 银行、语音助手、任何要求你"念一句话验证"的应用
  3. 与家人约定紧急暗语 → 选一个从未数字化过的短语,书面告知

AI创业 #数据安全 #生物特征 #语音克隆 #深度伪造 #隐私合规